據報導,輝達正全力研發至少達1兆參數的開源模型Nemotron 4,旨在降低對OpenAI等頭部客戶及雲巨頭的依賴。公司不僅通過回租服務器將雲服務算力承諾大幅增至280億美元,還組建了包括Mistral、Cursor等在內的「Nemotron聯盟」共建生態。輝達周二發佈300億參數、30億活躍參數的模型Nemotron 3.5 Lightning及開源模型路由庫NeMo Switchyard,分別主打高效智能體執行與多模型智能調度。戴爾宣佈擴大與輝達合作,將輝達官宣的這兩項技術納入Deskside Agentic AI,推動智能體向企業本地部署延伸。
輝達正在加速向開源AI模型的前沿競爭發起衝擊,試圖以此擴大GPU需求——儘管這一策略同時將其推入與自身客戶和投資對象正面競爭的微妙處境。
The Information本月11日周二報導稱,輝達目標是將Nemotron 4最大版本的性能打造至與全球頂尖開源模型比肩的水準。多名員工透露,該模型參數量預計至少達到一兆——約為其現有最大模型Nemotron 3 Ultra的兩倍。輝達生成式AI副總裁Kari Briski在一封郵件中表示,"輝達投資Nemotron,是因為我們相信每家企業、每個國家都需要可及的前沿開源模型。"
輝達當前的晶片需求高度集中於OpenAI、微軟、SpaceX等少數前沿實驗室和雲服務商,而上述機構正日益佈局自研AI晶片。Nemotron 4的推進旨在將需求基礎拓展至更廣泛的企業用戶群體,從而降低輝達對頭部客戶的依賴。AI模型評測機構Arena的首席執行長Anastasios Angelopoulos表示,"無論那家公司做出優秀的開源模型,輝達都是贏家。"